ICML 2026 | 突破极限!港大提出首个适配300+任务的持续学习架构,破解遗忘难题
ICML 2026 | 突破极限!港大提出首个适配300+任务的持续学习架构,破解遗忘难题人类可以在一生中持续学习新知识,而不会轻易遗忘已有技能。然而对 AI 模型而言,这恰恰是一道极具挑战性的难题:每当模型学习新任务时,参数更新往往会覆盖历史知识,产生经典的 “灾难性遗忘” 难题。持续学习(Continual Learning)正是为突破这一瓶颈而生的研究方向。
搜索
人类可以在一生中持续学习新知识,而不会轻易遗忘已有技能。然而对 AI 模型而言,这恰恰是一道极具挑战性的难题:每当模型学习新任务时,参数更新往往会覆盖历史知识,产生经典的 “灾难性遗忘” 难题。持续学习(Continual Learning)正是为突破这一瓶颈而生的研究方向。
Gradium 是一家总部位于巴黎、提供语音 AI 模型的初创公司,其对种子轮向包括 NVIDIA 在内的新投资者重新开放后,本轮融资总额现已达 1 亿美元,该公司周四表示 。这家初创公司是从法国 AI 实验室 Kyutai 分拆出来的(该实验室由 Niel 支持)。
流行的开源人工智能工具 Ollama 完成了 6500 万美元的 B 轮融资,由 Theory Ventures 领投,创始人兼首席执行官 Jeff Morgan 告诉 TechCrunch。Ollama 于 2023 年推出,帮助开发者在其个人电脑上运行开源权重的 AI 模型,让它们在数分钟内即可启动运行。
Base44 是一家 vibe-coding 平台,一年前被 Wix 以 8000 万美元收购。当时,这家公司成立还不到六个月,团队只有 8 个人。如今,Base44 开始推出自己的 AI 模型,帮助用户通过自然语言创建应用。
据外媒 The Information 报道:Meta 正在限制员工在 AI 模型构建中使用 Claude Code 和 Codex,原因是担心涉及模型蒸馏。 Meta 担心这些外部模型生成的内容,可能进入自家的训练数据或评测体系,从而引发所谓的模型蒸馏争议。
最近,我们都在关注旗舰级大模型的进步,其实本地运行的 AI 模型也迎来了重要的分水岭。
GlobalGPT 是一款很典型的 AI 套壳产品,一份订阅访问市面上几乎所有主流 AI 模型,目前全球累计用户超过 300 万,ARR 做到 1000 万美金。创始人李焕之,律师出身,2022 年开始连续创业,经历了 LegalDAO(Web3 法律社区)、LegalNow(AI 法律产品)的两次pivot后,在 2024 年初团队现金流只剩 1 个月时做出了 GlobalGPT。
几天前,OpenAI 用 AI 模型解决了一个关于点与点之间距离的数学问题,此前 80 年来这道题目一直未被完全攻克,消息一出一度被媒体刷屏。不过,没隔几天 16 位数学家站了出来,他们在荷兰莱顿大学发布了一份名为《莱顿宣言》的文件 [1]。
Bloomberg 曝出重磅消息:Trump 政府正在起草一份全新 AI 安全行政令。草案中没有强制模型测试条款,也不会要求前沿 AI 模型在发布前获得政府批准,取而代之的核心方向是「自愿合作」。从 Biden 时代的强制红队测试报告机制,到如今强调企业自愿参与网络防御——美国 AI 安全监管正在经历一次路线级别的转向。
这款 AI 工具名为 RetinaMind,利用视网膜图像训练 AI 模型,以百分比形式呈现对视网膜图像的置信度,通过这样的方式在疾病早期对 ASD 以及 ADHD 进行识别和诊断,准确率达 89%。不仅如此,该工具还可以帮助分析疾病基因机制(如 ABCA4)的潜在变化。